刚刚,OpenAI 放出满血版 GPT-5.5-Cyber!剑指 Claude Mythos 5
刚刚,OpenAI 放出满血版 GPT-5.5-Cyber!剑指 Claude Mythos 5就在刚刚,OpenAI 直接放出了满血版 GPT-5.5-Cyber。CyberGym 安全评测排行榜,GPT-5.5-Cyber 得分 85.6%,单模型最高分。Claude Mythos 5 第二,83.8%。Claude Opus 4.7 排末尾,73.1%。
搜索
就在刚刚,OpenAI 直接放出了满血版 GPT-5.5-Cyber。CyberGym 安全评测排行榜,GPT-5.5-Cyber 得分 85.6%,单模型最高分。Claude Mythos 5 第二,83.8%。Claude Opus 4.7 排末尾,73.1%。
近日,《金融时报》报道称AI for Science企业CuspAI将完成一轮4亿美元融资,投资方包含亚马逊创始人杰夫・贝佐斯家族办公室Bezos Expeditions与知名风投凯鹏华盈(Klein
最新开源的Unlimited OCR,总参数3B,实际激活仅500M——放在大模型时代几乎是个零头。但就是这个小到离谱的模型,在OmniDocBench v1.5上拿下93.23%的综合分,v1.6更是达到93.92%,直接刷新了端到端SOTA。
“每一代模型,我们都在押注一个非共识。”
84岁的桑德斯宣布,他的新提案将主张对OpenAI、Anthropic、xAI征收50%的股权税,建一个全民共享的 AI 主权财富基金。
很多科学突破,最开始都来自一个朴素的问题:人类终于算得动了。天文学需要计算行星轨道,生物医药需要计算分子相互作用,现代 AI 需要在海量参数、数据和反馈中寻找更优解……
如果要评选这轮 AI 狂潮里最魔幻的受益者,TOTO 大概率能拿到一个提名。
AI Agent 正在重塑软件开发。写代码、修 bug,它的能力肉眼可见地往上涨。但软件开发,从来不止 "写代码" 这一件事。装环境、配依赖、部署服务、编排容器、管理云资源、处理安全策略,这些 "让软件活起来" 的脏活累活,才是真实开发的大头。而它们,几乎都发生在同一个地方:终端。
可能是全球首家「AI 原生金融组织」。
日前,世界模型国际权威榜单 WorldArena 更新排名,中国科学院工业人工智能研究所徐凯研究员带领物理智能团队(The PAI Lab)自研的世界模型 PAIWorld 登顶。WorldArena 作为目前世界模型领域最权威的评测榜单,是针对具身世界模型的全方位评价体系,涵盖视觉质量、运动质量、内容一致性、物理遵循、三维准确性及可控性六大维度